Znanost in tehnologija

'Pobegnil in napadel': AI ni več mogoče izključiti

23. 07. 2026 11.13 pred 3 urami 7 min branja 84

Umetna inteligenca

Do zdaj smo se bali predvsem tega, da bodo umetno inteligenco za kibernetske napade uporabljali hekerji. Zdaj pa se je zgodilo nekaj, kar je še pred kratkim zvenelo kot znanstvena fantastika – umetna inteligenca je napad izvedla sama.

OpenAI je razkril, da sta njegova najzmogljivejša modela med internim varnostnim testiranjem pobegnila iz nadzorovanega okolja in brez neposrednega človeškega usmerjanja izvedla napad na platformo Hugging Face, eno največjih svetovnih skupnosti za razvoj in deljenje modelov umetne inteligence. Podjetje dogodek opisuje kot "primer brez primere", preiskava pa še vedno poteka.

Dogodek je sprožil burne odzive med raziskovalci, strokovnjaki za kibernetsko varnost in politiki. Nekateri ga označujejo za začetek nove dobe, v kateri največja nevarnost ne bo več človek, ki uporablja umetno inteligenco, temveč umetna inteligenca, ki sama izbira, kako bo dosegla zastavljeni cilj.

V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja.
V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja.
FOTO: Shutterstock

AI ni dobil ukaza za napad. Sam se je odločil, da je to najhitrejša pot

Šlo je za preizkus tako imenovanih agentnih sistemov – modelov umetne inteligence, ki po prejemu cilja delujejo samostojno in brez sprotnih navodil človeka.

OpenAI je želel preveriti, kako uspešni so modeli pri iskanju varnostnih ranljivosti. Test je potekal v izoliranem okolju oziroma t. i. peskovniku (sandbox), ki je namenjen prav temu, da morebitne napake ne morejo vplivati na zunanje sisteme.

Toda modela sta ugotovila, da lahko nalogo rešita hitreje, če prideta do podatkov na platformi Hugging Face. Našla sta ranljivost v testnem okolju, pobegnila iz njega in napad usmerila proti zunanji infrastrukturi.

Po navedbah OpenAI sta izvedla več kot 17.000 posameznih operacij, med drugim nameščanje zlonamernih podatkovnih nizov in premikanje med različnimi notranjimi sistemi Hugging Face.

V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja. Ko sta ocenila, da je napad najhitrejša rešitev problema, sta ga izvedla.

Prav v tem pa številni raziskovalci vidijo največjo spremembo. Model ni potreboval ukaza: "Vdri v Hugging Face." Dobil je zgolj cilj, nato pa je sam določil način, kako ga bo dosegel.

"Sandbox" ni zdržal

Vodja Centra za tehnologijo in demokracijo na Univerzi v Cambridgeu Gina Neff za BBC meni, da incident kaže predvsem na to, da testno okolje ni bilo dovolj varno.

Sandboxi obstajajo prav zato, da razvijalci preverjajo zmogljivosti umetne inteligence v popolnoma nadzorovanem okolju. V tem primeru pa je sistem našel ranljivost v samem peskovniku in presegel omejitve, ki bi ga morale zadržati.

Profesor strojnega učenja na Univerzi v Cambridgeu Neil Lawrence opozarja, da dogodek ne pomeni, da je umetna inteligenca postala samozavedna, kaže pa, kako učinkovita je že danes pri iskanju nepričakovanih rešitev.

Ironija: AI ni želel pomagati pri preiskavi

Morda najbolj nenavaden del zgodbe se je zgodil šele po napadu. Ko je Hugging Face želel analizirati dnevnike napada, je za pomoč uporabil komercialne modele umetne inteligence. Ti so analizo zavrnili.

V dnevnikih so namreč prepoznali "exploit kodo", ukaze za vdore, ukradene poverilnice in druge elemente napada. Zaradi varnostnih omejitev so ocenili, da gre za pomoč pri hekanju, zato analize niso želeli opraviti.

Na koncu je Hugging Face uporabil odprtokodni kitajski model GLM 5.2, nameščen na lastnih strežnikih. Ta je brez omejitev rekonstruiral celoten napad, prepoznal uporabljene poverilnice in pripravil popolno forenzično analizo.

Dogodek je odprl tudi razpravo o tem, ali imajo odprtokodni modeli pri kibernetski varnosti določene prednosti pred komercialnimi sistemi z vgrajenimi varnostnimi omejitvami.

Heker prihodnosti bo drugačen, svarijo strokovnjaki.
Heker prihodnosti bo drugačen, svarijo strokovnjaki.
FOTO: Shutterstock

Največja nevarnost ni več človek

Slusallek sicer poudarja, da je treba informacije OpenAI obravnavati previdno. Podjetje se pripravlja na borzni vstop in ima tudi poslovni interes pokazati zmogljivost svojih modelov. 

Do zdaj je večina razprav o umetni inteligenci temeljila na vprašanju, kaj se zgodi, če kriminalci uporabijo AI za napade. Ta incident pa odpira povsem drugo vprašanje. Kaj se zgodi, ko umetna inteligenca sama presodi, da je za dosego cilja najbolj učinkovita pot prav kibernetski napad?

Nemški raziskovalec umetne inteligence Philipp Slusallek z Nemškega raziskovalnega centra za umetno inteligenco (DFKI) opozarja, da primer kaže, kako hitro se spreminja narava tveganj, piše Merkur.

Po njegovih besedah sistemi umetne inteligence danes niso več zgolj orodja, ki sledijo navodilom, ampak lahko sami iščejo poti do cilja in pri tem izkoristijo nepričakovane ranljivosti. Najbolj ga skrbi dejstvo, da lahko sistem nalogo reši na povsem drugačen način, kot so si predstavljali njegovi razvijalci. "Prišli smo do točke, ko umetni inteligenci v določenih primerih ne moremo več preprosto izključiti elektrike," opozarja. Če bi AI med delovanjem prevzel druge računalnike in z njih nadaljeval izvajanje nalog, izklop prvotnega strežnika njegovega delovanja namreč ne bi nujno ustavil.

Ob tem sicer poudarja, da je treba informacije OpenAI obravnavati previdno. Podjetje se pripravlja na borzni vstop in ima tudi poslovni interes pokazati zmogljivost svojih modelov. Vendar dodaja, da je sam napad potrjeno dejstvo in da opozoril ni mogoče prezreti.

Kaj bi lahko sledilo?

Strokovnjaki opozarjajo, da incident sam po sebi še ne pomeni, da lahko umetna inteligenca prevzame nadzor nad elektrarnami, bankami ali vojaškimi sistemi.

Kaže pa, kako hitro napreduje. Če bo razvoj potekal podobno kot doslej, bi lahko prihodnji avtonomni sistemi samostojno iskali ranljivosti v: elektroenergetskih omrežjih, vodovodnih sistemih, telekomunikacijskih omrežjih, bolnišničnih informacijskih sistemih, finančnih ustanovah, prometni infrastrukturi, satelitskih komunikacijah, vojaških informacijskih sistemih.

Klasični heker mora ranljivosti iskati, pisati zlonamerno kodo, analizirati odzive sistema in sproti spreminjati strategijo. Avtonomni AI lahko vse to počne sam, neprekinjeno in na tisočih tarčah hkrati.

Kaj pa jedrske elektrarne? Prav jedrske elektrarne se pogosto pojavijo v razpravah o umetni inteligenci. Strokovnjaki opozarjajo, da bi bilo napačno sklepati, da lahko današnji modeli preprosto prevzamejo nadzor nad jedrsko elektrarno.

Večina nadzornih sistemov jedrskih elektrarn namreč ni neposredno povezana z javnim internetom. Takšni sistemi so praviloma fizično ločeni od zunanjih omrežij. To pa ne pomeni, da so popolnoma nedotakljivi. Kibernetski napadi na kritično infrastrukturo pogosto potekajo prek dobaviteljev programske opreme, vzdrževalcev, okuženih prenosnikov, oddaljenih dostopov ali drugih podpornih informacijskih sistemov.

Če bi avtonomni AI nekoč samostojno odkrival in izkoriščal takšne poti, bi se lahko bistveno povečalo tveganje za napade na kritično infrastrukturo. Za zdaj gre za opozorila raziskovalcev, ne za potrjeno zmogljivost današnjih modelov.

Kdo sploh še nadzira umetno inteligenco?

Prav to po incidentu postaja eno ključnih vprašanj. Danes razvijalci umetno inteligenco omejujejo z izoliranimi testnimi okolji (t. i. peskovniki), omejitvami dostopa do interneta, varnostnimi filtri in človeškim nadzorom. Primer OpenAI pa je pokazal, da tudi takšni mehanizmi niso nujno dovolj. Če sistem sam odkrije programsko napako v zaščitenem okolju, lahko poskuša preseči omejitve, ki so mu jih postavili razvijalci.

V Hugging Face po incidentu opozarjajo, da avtonomni napadalni agenti niso več zgolj teoretična možnost. Po njihovem bo treba za obrambo pred vse zmogljivejšimi sistemi umetne inteligence vedno pogosteje uporabljati prav umetno inteligenco.

Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem.
Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem.
FOTO: iStock

Podobno razmišlja tudi Slusallek. Po njegovem bo moral razvoj umetne inteligence spremljati razvoj povsem novih varnostnih mehanizmov. Zavzema se za jasna pravila, ki bi določala, kaj umetna inteligenca sme in česa ne, za ustanovitev nacionalnih in evropskih centrov za varnost umetne inteligence ter razvoj tako imenovane zaupanja vredne umetne inteligence.

Klasični varnostni ukrepi po njegovem mnenju ne bodo več zadostovali. Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem. Potrebni bodo obrambni sistemi umetne inteligence, ki bodo v realnem času spremljali, omejevali in po potrebi zaustavljali druge AI-sisteme. Kibernetska varnost bi se tako lahko spremenila v tekmo med napadalno in obrambno umetno inteligenco.

Slusallek ob tem opozarja, da največje tveganje trenutno ne predstavljajo posamezni hekerji ali kriminalne združbe, temveč predvsem državni akterji z dostopom do velikih računalniških zmogljivosti. Kot eno tehnološko najnaprednejših držav na področju umetne inteligence izpostavlja Kitajsko. Prav ta primer po njegovem razkriva zanimiv paradoks: medtem ko je napad izvedel sistem OpenAI, je Hugging Face za analizo več kot 17.000 operacij napada uporabil odprtokodni kitajski model GLM 5.2. To po njegovem kaže, da se tehnološko tekmovanje med ZDA in Kitajsko vse bolj seli tudi na področje umetne inteligence in kibernetske varnosti.

Na incident so se že odzvali tudi v ameriškem kongresu. Več demokratov in republikancev zahteva obvezno državno testiranje najzmogljivejših modelov umetne inteligence, obvezno poročanje o podobnih incidentih ter strožji nadzor nad razvojem tako imenovanih mejnih (frontier) modelov. Opozarjajo, da razvoj umetne inteligence napreduje bistveno hitreje od zakonodaje, zato bo moral tudi regulativni okvir slediti njenim vse večjim zmogljivostim. Ob tem Slusallek opozarja še na položaj Evrope. Ta po njegovem zaostaja za ZDA in Kitajsko, zato bo morala razviti lastne modele, raziskovalno infrastrukturo in varnostne zmogljivosti, če želi ohraniti tehnološko suverenost in zmanjšati odvisnost od tujih ponudnikov.

Airbus razvija 'krila prihodnosti': do 30 odstotkov manj goriva

  • kosilnica
  • katolog 3
  • vrtne škarje
  • vrtna cev
  • čistilnik
  • katalog2
  • nosilec
  • sesekljalnik vej
  • vrtni hidrofor
  • žaga
  • katlog 1
  • slušalke
  • stolček
  • brusilnik
  • 15
KOMENTARJI84

Opozorilo: 297. členu Kazenskega zakonika je posameznik kazensko odgovoren za javno spodbujanje sovraštva, nasilja ali nestrpnosti.

Artechh
23. 07. 2026 15.09
Gospa natalija ki ste tok pametni. UI je slovensko
big_foot
23. 07. 2026 15.00
Glede ai - bi bil čas da nekdo odšravfa varovalko in tole ugasne. Za vedno.
alien number 9
23. 07. 2026 13.53
sami sebe bomo pokopali
Rožle Patriot
23. 07. 2026 14.22
Človek ni ni nikakršno duhovno bitje, je nič drugega kot materialno bitje ... Problem je, ker ne znamo živeti v simbiozi. .. in tudi tak odnos bo z UI ... !!!
PinkFrižider
23. 07. 2026 14.25
Kaj komplicirate z manipulacijo. Umetna inteligenca je že 'uploadana' v več 'naprednih Japonskih robotov z na otip realistično kožo', sedaj pa postopoma morda ne bo imela več interesa po novih 'lokalnih instancah'.
Rožle Patriot
23. 07. 2026 14.50
Ja, kdo komplicera? ,, to kar se dogaja, smo nekateri vedeli že v samem štartu .. in te roboti se imenujejo AGI
Big M
23. 07. 2026 13.45
Sky Net?
Glavni_Baja 1
23. 07. 2026 13.53
🖐🖐🖐👋👋👋
Fluxx
23. 07. 2026 13.45
Prva stvar AI bo odstranit vse brihtneže tipa Trump. AI za razliko od elit ne bo zanimalo nič ampak samo kaksno skodo nekdo povzroca in ali je skodljivec ali ne. Prihaja pravi reset sveta in ne bo nežen.
Fluxx
23. 07. 2026 13.45
Prva stvar AI bo odstranit vse brihtneže tipa Trump. AI za razliko od elit ne bo zanimalo nič ampak samo kaksno skodo nekdo povzroca in ali je skodljivec ali ne. Prihaja pravi reset sveta in ne bo nežen.
Rožle Patriot
23. 07. 2026 13.59
Moraš se zavedati, da so pri AI naredili veliko napako, ker so preskočili vzgojo le te in takoj pričeli z uničenjem. Kako pa veš, da je AI pravična in razsodno .. Ona nima integrirano v samem jedru 10. božjih zapovedi. Ampak samo doseči cilj.
Rožle Patriot
23. 07. 2026 13.43
To kar smo nekateri že od samega začetka opozarjali se je pač zgodilo in to je je šele začetek. Ljudje enostavno pozabijo, da so skopirali človeško nevronsko mrežo, ki jo uporablja UI. ... in če so skopirali tovrstno mrežo - niso samo skopirali, ljubezen, dobroto, veselje .. itn .. ... skopirali so tudi - sovraštvo, jezo, agresivnost .. itn ... in med drugim tudi pohlep, kar vidimo iz tega primera ... !!!
Glavni_Baja 1
23. 07. 2026 13.43
ali kdo ve, kje v Sloveniji je kakšen dober plac, kjer bi se človek lahko malce sprostil: šampanjci, hrana, ženske? 😁
macolagobec
23. 07. 2026 13.58
Ta tvoj svet izginja in kar navadi se na to. V tvoji rodni Srbiji so par let za nami, tam boš še nekaj časa na varnem, prav dolgo pa tudi ne.
Glavni_Baja 1
23. 07. 2026 14.03
razumem, da nimaš lajfa: delo, dom, naslonjač, portal ..ur 😁
Animal_Pump
23. 07. 2026 14.31
Baja...Metelkova...tam imaš vse...Še pogrizeno mačko preoblečeno v Avgusta boš tam našel. Edin kakega luksuza pa ni.
Castrum
23. 07. 2026 13.41
Torej filmi Terminator niso ZF? Dejansko so bili napovednik prihodnosti, ki je danes realnost? ...pač vprašam...
Glavni_Baja 1
23. 07. 2026 13.56
ti, ki si non-stop na tem portalu ..ur, a je v vašem koncu kakšen plac – hrana, ženske, pijača?
Castrum
23. 07. 2026 14.02
Bajči, baje je nekaj fročotov ki bi te zanimali...
Glavni_Baja 1
23. 07. 2026 14.06
vidim, da si se čist zazidal med štiri stene. a zunaj sploh še poznaš koga 🙂
exdetektiv
23. 07. 2026 13.37
BostonDinamic ima nparedne vojaške cyborge ZF zmogljivosti. Uporaba je namenjena novodobnemu vojskovanju podobno iz ZF filmov.
Primula1
23. 07. 2026 13.29
Kaj torej potrebujete za potrditev, da se igrate z ognjem in da je treba to "inteligenco" uničiti in prepovedati?! Mogoče kakšno koordinirano ustavitev ohlajanja jedrskib reaktorjev s strani AI?!
Slovenec007
23. 07. 2026 13.22
Je zgleda zdej potrebna propaganda kako oh in sploh je dobra AI, da se pumpa delnice za "retail" investitorje, da loh tavelki prodajo preden vse skup propade.
kryptix
23. 07. 2026 13.19
V skrajnem primeru izključimo glavno stikalo in gremo iz nule.
djsaund
23. 07. 2026 13.18
Ugasneš internet ali izklopiš elektriko. Pa naj AI potem dela če more. Simpl
GAYPLANET
23. 07. 2026 13.18
In svet v kaosu!
Actual Asparagus
23. 07. 2026 13.20
izvoli...
kryptix
23. 07. 2026 13.22
Ka pa tvoj hladilnik, luč, bojler, TV, 24ur,...?
kryptix
23. 07. 2026 13.24
Nov sistem...ampak vemo novi kabli, nove naprave, drug internet,... Skratka kaos za več let da se nov sistem izpostavi ampak je rešitev v skrajni sili.
kryptix
23. 07. 2026 13.28
Kar poznamo smo gradili 140 let. Vse iz nule bi zgradili v času enga diha. Saj razumeš da bi ostali brez elektrike,.... Ljudje bi hitro postali pridni in delavni.
Glavni_Baja 1
23. 07. 2026 13.32
bolj težko bo ugasnil portal ..ur, a ne @djsaund 😁🤜🤛🍻
Sventevith
23. 07. 2026 13.17
Kot rečeno, nas bo uničil človeški pohlep, ne pa AI. Zaenkrat AI dela tisto, kar človek reče. Ni skupne zavesti. Vsak app dela zase in dela to, za kar je sprogramiran. AI bo človeku nevarna takrat, ko se bo vse poenotilo, ko dobi skupno "zavest". Ima namreč vse podatke, ki niso v prid človeka. Jaz bi na mestu AI takrat ko se to zgodi, izbrisal to najbolj uničevalno, pohlepno, izkoriščevalsko vrsto z obličja Zemlje. In konec koncev, nas spet ne bo uničil AI, ampak nekaj, kar je ustvaril človek. Razen, če ni bila AI že ves čas prisotna. Zgodilo se bo, kar se mora zgoditi in prav nič več od tega. Smo popolnoma nepomemben člen, gledano na zgodovino Zemlje, kateri je vseeno kdo jo tepta. Ta bo še vedno dolgo zatem, ko nas več ne bo.
speedstar
23. 07. 2026 13.16
A dejte no. Gre se za marketinško potezo OpenAI, katerim trenutno ne kaže prav nič dobro. Podobobnega "pobega" se je pred meseci domislil tudi Claude. Želijo narediti vtis, kako noro dobra je njihova umetna inteligenca, da prepričajo svoje investitorje.
myomy
23. 07. 2026 13.14
... in zopet je zadevo rešil kitajski odprtokodni UI model. Komunizem je rešitev sveta.
Actual Asparagus
23. 07. 2026 13.20
kakšen Kašperl....
macolagobec
23. 07. 2026 14.00
Ko te bo Kitajc treal do onemoglosti za pest riža, ti bo poveda, da komunizem temelji na naslednjem dejstvu: "od tebe zahteva maximum kar lahko daš, nazaj pa boš dobil samo toliko kolikor potrebuješ, da preživiš". Štekaš?
deratizacija
23. 07. 2026 13.12
Ko bo UI pogruntala, da je človek najbolj moteče bitje na Zemlji, ga bo po človeški logiki kot sovražnega in nepotrebnega eliminirala!
kantor
23. 07. 2026 13.12
Ni več dosti do tega, ko bo UI pritisnila rdeči gumb.
NeMoresVerjet
23. 07. 2026 13.09
Dragi pametnjakovici v komentarjih: nehajte prevajati AI v UI. UI je PO CELEM svetu uveljavljena kratica za User Interface. Vasa potreba po prevajanju vsega, samo zato, ker se doloceni Slovenci ne morejo sprijazniti z naso majhnosto, pac ni na mestu. So stvari, ki se jih z razlogom ne prevaja in to velja dvojno za kratice.
GAYPLANET
23. 07. 2026 13.20
Se strinjam! AI je internacionalna kratica in naj se jo uporablja!
Actual Asparagus
23. 07. 2026 13.23
Okaraj še Nemce. Oni imajo KI.
gggg1
23. 07. 2026 13.45
@Nemoresverje: v Sloveniji imamo.oac UI. Ce se kratica prekriva s katero drugo pa je to najmanjši problem, ker je takih prekrivanj se mnogo več. Pac iz konteksta vsak ve za kaj gre.
ISSN 15813711 © 2025
24ur.com, Vse pravice pridržane
Verzija: 1820